AI资讯新闻榜单内容搜索-AI

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: AI
过程奖励模型也可以测试时扩展?清华、上海AI Lab 23K数据让1.5B小模型逆袭GPT-4o

过程奖励模型也可以测试时扩展?清华、上海AI Lab 23K数据让1.5B小模型逆袭GPT-4o

过程奖励模型也可以测试时扩展?清华、上海AI Lab 23K数据让1.5B小模型逆袭GPT-4o

随着 OpenAI o1 和 DeepSeek R1 的爆火,大语言模型(LLM)的推理能力增强和测试时扩展(TTS)受到广泛关注。然而,在复杂推理问题中,如何精准评估模型每一步回答的质量,仍然是一个亟待解决的难题。传统的过程奖励模型(PRM)虽能验证推理步骤,但受限于标量评分机制,难以捕捉深层逻辑错误,且其判别式建模方式限制了测试时的拓展能力。

来自主题: AI技术研报
9751 点击    2025-04-14 14:39
解秘阿里 AI 战略:从未发布,但已开始狂奔

解秘阿里 AI 战略:从未发布,但已开始狂奔

解秘阿里 AI 战略:从未发布,但已开始狂奔

阿里巴巴可能看清楚了,自我迭代,不仅是靠用户价值和创业精神的回归,更需要的,是一场生产力革命。

来自主题: AI资讯
7052 点击    2025-04-14 14:34
10万奖金×认知升级!OceanBase首届AI黑客松广发英雄帖,你敢来么?

10万奖金×认知升级!OceanBase首届AI黑客松广发英雄帖,你敢来么?

10万奖金×认知升级!OceanBase首届AI黑客松广发英雄帖,你敢来么?

从 ChatGPT 引发认知革命到 GPT-4o 实现多模态跨越,AI 技术的每次跃迁都在印证一个底层逻辑 —— 数据质量决定智能高度。而今,这场 AI 浪潮正在反哺数据库领域,推动其从幕后走向台前,完成智能时代的华丽转身。

来自主题: AI资讯
10921 点击    2025-04-14 14:28
谷歌追赶 OpenAI 的“一百天”

谷歌追赶 OpenAI 的“一百天”

谷歌追赶 OpenAI 的“一百天”

这家科技巨头通过昼夜奋战、大举裁员以及非常规手段,实现了技术代差的快速弥合。

来自主题: AI资讯
5922 点击    2025-04-14 14:22
更长思维并不等于更强推理性能,强化学习可以很简洁

更长思维并不等于更强推理性能,强化学习可以很简洁

更长思维并不等于更强推理性能,强化学习可以很简洁

今天早些时候,著名研究者和技术作家 Sebastian Raschka 发布了一条推文,解读了一篇来自 Wand AI 的强化学习研究,其中分析了推理模型生成较长响应的原因。

来自主题: AI技术研报
9171 点击    2025-04-14 14:17
12名OpenAI前员工公开支持马斯克诉讼,指责OpenAI重组违反非营利使命

12名OpenAI前员工公开支持马斯克诉讼,指责OpenAI重组违反非营利使命

12名OpenAI前员工公开支持马斯克诉讼,指责OpenAI重组违反非营利使命

近日,一场关于 OpenAI 未来走向的激烈纷争正在上演。4 月 11 日,12 名 OpenAI 前员工联合提交了一份法律简报,明确表态支持埃隆·马斯克对 OpenAI 提起的诉讼,这场诉讼的核心在于 OpenAI 从非营利组织向营利性实体的转型。

来自主题: AI资讯
10944 点击    2025-04-14 13:51
GitHub中国IP访问崩了又复活!OpenAI API新政恐锁死GPT-5?

GitHub中国IP访问崩了又复活!OpenAI API新政恐锁死GPT-5?

GitHub中国IP访问崩了又复活!OpenAI API新政恐锁死GPT-5?

GitHub中国区昨日突然访问受限,官方最新回复:只是一个配置失误导致的,现已全面恢复。与此同时,OpenAI推出API「已验证组织」新政,全球开发者想用前沿模型,得先过这关!

来自主题: AI资讯
7027 点击    2025-04-14 11:55
Cursor 迎来了强大的对手,Augment Code实测

Cursor 迎来了强大的对手,Augment Code实测

Cursor 迎来了强大的对手,Augment Code实测

根据官方介绍,Augment Agent 是首个转为大型代码库工作的专业软件工程师设计的 AI 编码助手,上下文支持 200K ,也就是 20 万的 token 啊。

来自主题: AI资讯
11554 点击    2025-04-14 11:10
强化学习带来的改进只是「噪音」?最新研究预警:冷静看待推理模型的进展

强化学习带来的改进只是「噪音」?最新研究预警:冷静看待推理模型的进展

强化学习带来的改进只是「噪音」?最新研究预警:冷静看待推理模型的进展

尽管这些论文的结论统统指向了强化学习带来的显著性能提升,但来自图宾根大学和剑桥大学的研究者发现,强化学习导致的许多「改进」可能只是噪音。「受推理领域越来越多不一致的经验说法的推动,我们对推理基准的现状进行了严格的调查,特别关注了数学推理领域评估算法进展最广泛使用的测试平台之一 HuggingFaceH4,2024;AI - MO。」

来自主题: AI技术研报
6486 点击    2025-04-13 15:59